Ejecutar modelos de inteligencia artificial avanzados directamente en el ordenador sin depender de servidores externos ya es posible. AMD ha mostrado las primeras pruebas de rendimiento del nuevo modelo Muse Glimmer 30B, desarrollado por Meta Superintelligence Labs. Durante los ensayos, una tarjeta gráfica AMD Radeon™ AI PRO R9700 alcanzó una velocidad de hasta 53 tokens por segundo. Asimismo, el procesador AMD Ryzen™ AI Max+ 395 logró procesar hasta 24 tokens por segundo en un equipo configurado con 128 GB de memoria del sistema.
Muse Glimmer 30B es un modelo de código abierto publicado bajo la licencia Apache 2.0. Dispone de 30.000 millones de parámetros enfocados en flujos de trabajo con agentes autónomos. A diferencia de un asistente tradicional, este sistema gestiona tareas complejas divididas en múltiples pasos. La arquitectura conserva la memoria entre sesiones, utiliza herramientas locales, corrige sus propios errores tras un fallo imprevisto y protege la privacidad al procesar la información dentro de la máquina.
Optimización en Windows con llama.cpp y soporte para desarrolladores
Las mediciones de rendimiento se realizaron sobre el sistema operativo Windows 11. Para ello se utilizó el proyecto de código abierto llama.cpp junto con el motor gráfico Vulkan y la técnica de decodificación especulativa dFlash. Este lanzamiento complementa los avances de la compañía en el sector del software. Hace poco te contamos que Meta presentó recientemente su entorno de desarrollo Muse Code para la terminal.
El despliegue de esta IA en el equipo resulta accesible mediante la aplicación LM Studio. Los ordenadores equipados con más de 32 GB de memoria VRAM o memoria gráfica variable pueden descargar y ejecutar el modelo en pocos minutos. Además, el programa permite compartir el servicio en la red local. Esta función facilita conectar la IA con agentes autónomos como Hermes Agent u OpenClaw mediante interfaces compatibles con los estándares de OpenAI y Anthropic.
Para la integración en software de terceros, los creadores de aplicaciones cuentan con la herramienta Lemonade. Esta utilidad consiste en un archivo ejecutable empaquetable de solo 4 MB. El programa detecta automáticamente el hardware de la máquina y selecciona el motor óptimo para procesadores Ryzen AI o tarjetas gráficas Radeon. De este modo, los desarrolladores pueden ofrecer funciones privadas de automatización e investigación sin obligar al usuario a realizar configuraciones técnicas complejas.
Te interesa 👉 Los mejores procesadores que puedes comprar
La combinación de componentes de hardware dedicados y ecosistemas de software abiertos consolida la tendencia de los ordenadores con agentes locales. Esta arquitectura elimina los costes recurrentes por consumo de tokens en servicios externos. Al mismo tiempo, garantiza que los archivos, contraseñas y credenciales de trabajo permanezcan bajo el control exclusivo del usuario.